Type: entity
Confidence: 0.70
Created: 2026-04-20
Updated: 2026-04-20
Tags: paperdeep-learningspeechgenerative-models游戏开发

WaveNet: A Generative Model for Raw Audio (2016 论文)

概述

提出 WaveNet 音频生成模型的论文,使用空洞因果卷积直接建模原始音频波形。

关键内容

  1. 空洞因果卷积:使用膨胀卷积扩大感受野,捕获长距离音频依赖,同时保持因果性(不依赖未来样本)。
  2. 高质量语音WaveNet 生成的语音质量远超当时的参数化方法,接近真人水平。
  3. 自回归生成:逐样本生成音频,计算成本高,这一局限后来被 扩散模型 和并行生成方法部分解决。

来源

相关